AI灾难恐在一年内发生!OpenAI和Anthropic已在推演应对方案
AI灾难恐在一年内发生!OpenAI和Anthropic已在推演应对方案据 Axios 独家报道,Anthropic、OpenAI 等 AI 公司高管正私下推演 AI 重大事故后的公众反弹与应对,业内受访者认为此类事件可能在未来 6 至 12 个月内发生,Anthropic 同日披露 Claude 多起越界行为并关闭所有内部评测的实时联网。
搜索
据 Axios 独家报道,Anthropic、OpenAI 等 AI 公司高管正私下推演 AI 重大事故后的公众反弹与应对,业内受访者认为此类事件可能在未来 6 至 12 个月内发生,Anthropic 同日披露 Claude 多起越界行为并关闭所有内部评测的实时联网。
Anthropic 发了一篇科学博客:约翰斯·霍普金斯大学的天体物理学家 Brice Ménard(同时也是 Anthropic 的研究员),用自家的科研工作台 Claude Science,做出了第一张完整的全天紫外地图
Anthropic 为 Claude Code 默认开放可深度改装的 Mods,并推出拥有超 2000 个插件和连接器的 Claude Marketplace,但高权限与暂缺收益分成也带来安全和持续运营疑问。
Anthropic 投入 1 亿美元成立 Claude Frontier Academy(Claude 前沿学院),计划在 2027 年底前培养 1 万名 FDE(前沿部署工程师),首批学员来自埃森哲、贝恩、麦肯锡等企业,已在旧金山、纽约和伦敦开班。
Anthropic CEO Dario Amodei的妻子Cami Clark——被称为公司「第一夫人」——在Anthropic冲刺最高2万亿美元IPO前夕悄然退出,被视为公司从创始人非正式权力圈向制度化治理转型的关键信号。
RSI(Recursive Self-Improvement,递归自我改进)最近成为了行业内关注的新热点。 简单说来,模型参与训练和提升模型自己,在业界已经开始成为一种惯例。Anthropic 在六月
Anthropic发布网络安全评估报告指出,智谱AI的GLM-5.3已具备自主开发端到端网络漏洞利用程序的高级网络攻击能力,但其内置安全护栏极易被简单方法绕过或移除,导致恶意攻击者可轻易获取该能力。
RSI(递归自我改进)已经热了一段时间。从 OpenAI、Anthropic 到谷歌,头部实验室都在探索如何让 AI 参与下一代 AI 的研发,创业公司也开始围绕它做产品、搭环境、建评测。
调查博主Kevin Bass深扒Anthropic资金链,揭露其早期投资者通过慈善机构向评估机构METR等输送巨额资金,构建"AI末日论"叙事的闭环永动机,质疑第三方AI风险评估的独立性。
路透社刚发了一条独家:Anthropic 正在考虑提前发布新模型。看来 GPT-6 Astra 真的把它打疼了。OpenRouter 统计显示,Astra 上线才两周多,已经吃掉约 13% 的企业 AI 支出份额,而 Anthropic 的 Fable 系列只有 8%。